Benchmarking Speech Recognition Models for Medical Consultations in Latin American Spanish: A Comparative Evaluation with Fine-Tuning
본 연구는 라틴 아메리카 스페인어 의료 상담을 대상으로 10개의 음성-텍스트 변환 모델을 벤치마킹하였으며, Whisper Large v3를 미세 조정하는 것이 기존 버전을 능가하지는 못했으나 주요 지표에서 다른 오픈 소스 및 폐쇄형 모델들보다 우수한 성능을 보였다는 점을 발견하여, 이를 해당 맥락에서 AI 의료 기록 작성을 위한 최적의 오픈 소스 솔루션으로 확립하였다.